Perplexity 推出便携式 AI 计算机,主打本地优先与零 token 计费
Perplexity 发布便携式 AI 计算机,作为其智能体平台 Computer 的本地优先版本,可直接在 NVIDIA DGX Spark 上运行智能体工具链、编排器、规划器和后训练模型。系统将本地模型、推理引擎、工具沙箱与应用连接器打包,设备端处理的任务不产生按 token 计费成本;如需实时联网或更强推理,编排器会征求用户同意后,将单一步骤发送至 15 个以上云端模型之一。

Perplexity 发布便携式 AI 计算机,作为其智能体平台 Computer 的本地优先版本,可直接在 NVIDIA DGX Spark 上运行智能体工具链、编排器、规划器和后训练模型。系统将本地模型、推理引擎、工具沙箱与应用连接器打包,设备端处理的任务不产生按 token 计费成本;如需实时联网或更强推理,编排器会征求用户同意后,将单一步骤发送至 15 个以上云端模型之一。

小米公开 AI Cube 工程原型机,主打 160GB 统一内存,并将其与英伟达 DGX Spark、苹果 Mac Studio 放在同一竞争坐标。报道指出,全球 DRAM 合约价今年第一季季增约 90% 至 95%,第二季预估再增约 58% 至 63%,内存短缺正推高桌面 AI 设备成本。AI Cube 目前仍未公布售价与量产时间,小米能否发起价格竞争,仍取决于内存供应。

英伟达发布开源 AI 模型 NVIDIA Ising Calibration 1.5,用于自动分析量子处理器诊断数据并生成调校方案,推动量子计算机校准流程自动化。该模型面向量子计算校准场景设计,在 QCalEval 基准测试中,零样本推理平均领先同规模开源模型约 10%,结合上下文学习时较上一代提升约 86.5%。模型参数规模为 310 亿,支持数据中心 GPU 与单张消费级 GPU 部署。

作者称,用 2999 美元的 NVIDIA DGX Spark 替代每月约 1900 美元的云端 GPU 租用后,首年可把约 2.2 万美元留在业务内。核心在于 128GB 统一内存与本地部署能力。

以太坊创始人Vitalik Buterin宣布彻底脱离云AI,采用完全本地化、沙盒化的AI系统。他警告约15%的AI代理技能含恶意指令,并分享了基于Nvidia 5090 GPU和Qwen3.5模型的私有LLM部署方案。

Vitalik Buterin称,云端AI正带来隐私泄露、恶意指令和未授权操作风险,主张采用本地推理、本地存储、沙箱隔离与人工确认的本地优先方案。

Vitalik Buterin提出本地部署私有大模型方案,强调本地推理、设备端存储与沙箱隔离,以降低数据泄露和未授权访问风险,并披露多款硬件实测表现。

以太坊创始人Vitalik Buterin公布了部署本地私有大语言模型(LLM)的计划,强调隐私与安全。他测试了搭载NVIDIA 5090、AMD Ryzen AI Max Pro和DGX Spark等硬件,并分享了Qwen3.5模型的性能数据,其中5090达到90 tokens/秒。
